Long Ouyang
概述
OpenAI 研究员,InstructGPT 论文的第一作者,推动了大语言模型的人类偏好对齐研究。
关键内容
- InstructGPT 论文(2022):作为第一作者发表《Training language models to follow instructions with human feedback》,展示使用 RLHF(基于人类反馈的强化学习)对齐大语言模型。
- RLHF 流程:通过监督微调、奖励模型训练、PPO(近端策略优化) 优化三步流程,使模型输出更符合人类偏好。
- ChatGPT 前身:InstructGPT 是 ChatGPT 的直接技术前身,其对齐方法成为大语言模型部署的标准实践。
来源
- ai_papers_timeline.md — 2022 年时间线条目
相关
- OpenAI — affiliated_with
- InstructGPT — contributed_to
- PPO(近端策略优化) — applied
- RLHF — contributed_to